Liquid AI发布面向视觉语言模型LFM2.5-VL-3B的实验性DSpark草稿模型,通过推测解码在不改变输出质量的前提下提升推理速度:端侧解码最高加速3.13倍、H100上2.66倍,端到端最高2.62倍和2.27倍;草稿模型新增2.8亿参数,仅增加8.9%参数量,并首日支持llama.cpp、MLX-VLM和SGLang。